메뉴

#AI 학습데이터

WR
Wired AI • 14일 전
IMP 8

메타, AI 학습·안면인식 데이터에 사진 불법 사용으로 집단소송

일리노이·캘리포니아 주민들이 메타를 상대로 집단소송을 제기, 페이스북·인스타그램 사진을 동의 없이 생체정보로 추출해 미공개 안면인식 시스템 '네임택(NameTag)'과 생성형 AI(Emu, Muse Image) 학습에 사용했다고 주장했습니다. 원고측은 일리노이 생체정보보호법(BIPA)에 따라 위반당 최대 5,000달러의 배상을 청구하며, 집단소송 대상이 수백만 명에 달할 수 있습니다.

메타 안면인식 생체정보
HN
Hacker News • 39일 전
IMP 7

구글, 파산 항공사 스피릿 데이터를 경매에서 1,000만 달러에 낙찰받다

2026년 5월 영구 운항 중단 후 청산 절차에 들어간 미국 저가 항공사 스피릿의 데이터가 경매에 부쳐졌고, 구글이 1,000만 달러에 낙찰받았습니다. 구글은 1억 건의 이메일, 3천만 건 이상의 녹음 고객 상담 전화, Teams·Oracle·SAP 데이터 등 방대한 자료를 확보했으며, AI 서비스 향상 목적이라고 밝혔습니다. 데이터는 비식별화되었고 구글은 개인정보(PII) 발견 시 삭제하겠다고 약속했지만, 완전한 안전성에 대한 의문은 남습니다.

구글 AI 학습데이터 데이터 프라이버시
TC
TechCrunch AI • 39일 전
IMP 7

아마존, AI 학습용으로 희귀 도서 절단·파괴 논란

아마존이 희귀 도서를 대량으로 구매해 책등을 잘라내 스캔한 뒤 AI 모델 학습 데이터로 활용하는 것으로 드러났습니다. 404 미디어가 추적 장치를 넣은 희귀 서적이 라스베이거스 아마존 시설에 도착하는 것을 확인했습니다. 인터넷에서 구할 수 없는 절판 도서는 2022년 이전 출간으로 AI 생성 텍스트가 섞이지 않아 모델 붕괴(model collapse)를 피할 수 있는 귀중한 학습 데이터로 주목받고 있습니다.

아마존 AI 학습데이터 저작권